這二十幾天寫下來,介面切來切去、規範改來改去,都是在解決「我自己」(技術人)怎麼用得更順的問題。但有個場景一直放在心裡沒處理:回家的時候,當長輩問「AI 到底是什麼?是聊天機器人嗎?你在忙什麼?」
我發現自己講不出一段對方聽得懂又不失真的話。
講太淺,變成「就是問問題它會回答」,對方就當作是聊天機器人;講太深,第三句話出現「模型」、「上下文」,注意力就消失了。那條界線很難抓,而且抓不到的原因不在技術,在於我太熟悉這些詞,已經失去判斷哪些詞是門檻的能力。
所以今天做的事情很單純:跟 Claude 一起做一份可以真的拿去講的簡報,對象設定成完全沒碰過 AI 的長輩。我把想講的內容跟每一段的重點先打成一份需求檔(Day29-需求.txt),再整包丟給 Claude Code(Opus 5、Medium)去做,二十六頁一次生出來,設計稿跟 PowerPoint 兩種格式一起輸出。
一開始列的大綱是二十四頁,過程中被加到二十六頁;加的那兩頁,剛好就是我原本看不見的那兩個洞。真正有價值的,是排大綱這個過程逼我看到自己講法的破洞。
完整簡報檔可以在這裡取得:Day29-初入AI-LLM世界-簡報.pptx。
第一頁就決定了後面二十五頁對方要不要繼續聽。這裡刻意不用「類神經網路」、「參數量」這種詞,改成兩個對照:AI 是大範疇,LLM 是其中一種,而且是現在最常被講到的那一種。

「讀過非常多書、記憶力很好、但偶爾會記錯細節的助理」這個比喻是整份簡報裡最重要的一句話。它同時交代了能力來源(讀過很多)跟侷限(會記錯),後面講幻覺的時候可以直接回頭引用,不用再重新鋪陳一次。右邊那張卡片則是把抽象名詞接回生活經驗:ChatGPT 其實就是 LLM 的外殼,只是包裝成一般人用得到的樣子。
接下來兩頁是時間軸。原本想跳過歷史直接教操作,但我知道用歷史脈絡激起回憶的重要性,長輩對「這東西是不是又一個一年就消失的流行」的疑慮很重,講清楚它已經累積十幾年,接受度會差很多。

2012 年以前用一行帶過就好,重點放在 AlexNet、AlphaGo、Transformer 這條線上。AlphaGo 是這一頁的錨點,因為那是多數人第一次在新聞上真的注意到 AI,講到那格會看到對方點頭。有共同記憶的那一格,就是整條時間軸的施力點。(實際上我在講給爸媽聽的時候,他們對這件新聞的反應很大)

第二條時間軸從 2022 年 11 月切開,講的是「從工程師的玩具變成一般人的工具」。這頁的收尾寫「重點不是記住年份,是感受到這件事一直在加速」,是刻意留的,因為長輩最常見的反應是「那我現在學,會不會馬上就過時」。
第二段的目的很實際:讓對方知道要去哪裡註冊,以及不要被隨便一個 App 騙進去。

六個名字配六個網址,沒有多餘的說明。這頁的功能是「照著念、照著打」,所以網址必須大到在螢幕上看得清楚。

每張卡只留四件事:名字、公司、一句特色、適合誰。
寫成「已經在用 Google 全家桶的人」、「常用 Word/Excel/Outlook 的人」,對方就能自己對號入座,這比我替他選一個好。

講三件可驗證的事:資料可能存在中國境內、依當地法規需配合調閱、敏感議題的回答會被引導。
這一頁的風險跟前面幾頁不一樣。用錯模型頂多是答案品質差一點,這裡講的是資料流向,病歷、保單丟進去之後就收不回來。而且這些服務名字看起來都很正常,介面也是繁體中文,還免費。實務上不用記名字,回到第 4 頁那六個網址進去就好,對非技術背景的使用者,白名單永遠比黑名單好用。

原本猶豫要不要放這頁,覺得跑分榜有點太工程師視角。留下來的理由是:與其講「現在 X 最強」讓對方記一個半年後就過期的答案,不如給一個之後可以自己查的地方。

里程碑這頁跟第一段的時間軸有點重疊,差別在這頁挑的是「社會層面被認可」的事件:AlphaGo、ChatGPT 上線、各國開始討論監管、AlphaFold 拿諾貝爾化學獎。

上下兩條平行時間軸,上面 ChatGPT、下面 Claude。這頁的重點寫在最底下那行:版本號不用背,因為現在用的版本半年後可能就換代。這句話是講給「怕學了會過時」的人聽的,真正的答案是連 AI 自己都在換代,所以放輕鬆。
原本的大綱從「AI 是什麼」直接跳到「怎麼問問題」,中間少了一段。想像一下實際場景:長輩聽完前面九頁,點頭說好,然後拿起手機,接著就卡住了,因為不知道要下載哪個、要不要辦帳號、辦帳號要不要記密碼。

所以補了這一頁,四個步驟:去哪裡找、用 Google 或 Apple 帳號登入就好(不用再記一組新密碼,這點對長輩很關鍵)、不會打字可以按麥克風用說的、先用免費版。
打字對很多長輩是真正的門檻,一句話要找十幾個注音,還沒問完就放棄了。語音輸入把這個門檻整個拿掉,而且現在辨識率好到可以直接講台語夾雜國語。
這一頁的位置也刻意排在「介紹完有哪些選擇」之後、「教怎麼問」之前,順序才連得起來。
這是整份簡報的核心,八頁。

三個例句都刻意挑長輩生活裡真的會遇到的事:血壓飲食、水電費帳單、可疑的 LINE 訊息。這比「幫我寫一封求職信」貼近得多。

分成「憑記憶回答」跟「上網查完再回答」兩種,是為了解釋一個很常見的困惑:為什麼同一個 AI 有時候答得出今天的天氣,有時候卻說自己不知道最近的事。理解這個差別之後,就知道問時效性問題時要主動補一句「上網查一下最新的」。

記憶功能這頁我把好處跟風險放在同一頁、同樣大小的兩張卡片,沒有讓好處那張比較大。提過一次有什麼慢性病,之後問飲食建議會自動考慮進去,這很方便;但同一個機制也意味著講出去的東西會留在雲端帳號裡。

幻覺、使用者偏好、上下文限制,三個一起講。
幻覺最難講的地方,在於它不是「答不出來」,而是「答得很有自信但內容是錯的」,而且錯得愈具體愈危險。所以簡報上把它跟第一頁那個比喻接回去:讀過很多書但偶爾記錯細節的助理,記錯的時候不會特別提醒。
第二點「使用者偏好」是我覺得最少被提醒、但對長輩最危險的一項。AI 會慢慢順著對話者原本的思考方式回答,用久了很容易產生「連 AI 都同意我」的錯覺,但那不是驗證,那是回音。
第三點則有一個很實用的操作建議:聊太久、貼太多資料之後,開一個新對話反而比在舊對話裡繼續拉扯清楚。很多人卡在「明明前面講過了它怎麼又忘記」,以為是它壞掉,其實只是這段對話已經太長。

開放式跟敘述式的對照,用同一個情境寫成兩句實際的話:「幫我想幾個週末台北室內景點」對上「想 3 個台北室內景點,帶 70 歲長輩,輪椅可進出、不用爬樓梯」。兩句並排,不用解釋就看得出差在哪。

背景、限制條件、呈現方式、直接改。四步驟裡最有價值的是第四步:不滿意的時候講哪裡不對就好,不用整句重問。

AI 對齊(Alignment)跟 AI Harness Engineering 這一頁,是整份簡報裡唯一標上「進階」的內容。做的時候掙扎過要不要拿掉,對完全沒碰過 AI 的人來說門檻明顯高於其他頁。
最後保留,但要求自己一定要配一句白話收尾:「同樣一顆大腦,裝在不同的殼裡,個性和謹慎程度會不一樣。」
留著的理由是:不講這段,很容易讓人以為 AI 的回答是「電腦算出來的客觀答案」,那後面那句「不要全信」就只剩客套的免責聲明。

RULE 跟 SKILL 這頁做了一個轉譯:把平常在 Claude Code 裡用的規則與技能概念,對回消費版 App 裡的「自訂指示」跟「自訂 GPT/Gemini Gem」。概念是同一個:與其每次重講一次習慣,不如設定一次之後都記得。寫這兩頁的時候特別有感,畢竟這二十幾天有一半的時間都在跟自己寫的規則角力。

這一段是整份簡報的「有感」環節。前面講的都是問答,這裡講的是產出。對長輩來說,看到一份可以下載打開的 Excel 從對話框裡跑出來,衝擊比什麼都大。對關注股市的長輩來說,好像又方便了一些xD
會把這段放在後面,是因為它需要前面的鋪陳。一開始就做這個,容易變成「很厲害但跟我無關」的表演;等到對方已經知道它怎麼回答、也知道它會出錯,再看到它產出檔案,接受的方式會不一樣,那是一個實際可以使用的「工具」。

題目選保健食品是刻意的:這是長輩自己會關心、家裡也真的有一整櫃的東西。欄位設計成品項、建議劑量、服用時機、注意事項,其中「注意事項」那欄最有價值:魚油與抗凝血藥物、B 群與睡眠、益生菌與抗生素間隔,這些是平常買回來根本不會去查的資訊。

筆記本這類功能的價值,在於把回答的範圍鎖在自己丟進去的資料裡,而不是整個網路。這頁跟前面講幻覺那頁是配套的:知道 AI 會答錯之後很自然會問「那要怎麼辦」,把範圍縮小就是一個實際的答案,要查證也只需要翻那幾份文件。

影片轉逐字稿這頁配的情境是健康講座,一小時的影片先讓 AI 整理重點,需要細節再回去看。(其實 Claude 這邊忽略了長輩更想關心股票XD 前幾天把總經指標做成網頁其實有個原因也是為了長輩方便看)

習慣邊做事邊聽廣播的長輩特別對味(例如我媽)。

從零生成跟修改既有檔案,在使用心態上差很多。前者像是「AI 幫我做了一份」,後者是「我的東西被改好了」,後者的門檻感低很多,也比較容易變成日常習慣。

三句話收尾:多用但不要全信、跟用 Google 一樣要小心、以後會愈來愈整合所以現在開始熟悉。第二句是刻意的類比。長輩對「Google 到的東西不一定對」這件事已經有經驗,把 AI 掛在同一個既有認知上,比從頭建立一套新的警覺容易得多。

最後這頁是整份簡報最晚才加進去、Claude 認為最該講的一頁。
三件事:身分證字號、銀行帳號、提款密碼、健保卡號不要貼進任何 AI 聊天視窗;深偽的語音跟影片已經足以偽造「家人急需用錢」的求救;反過來,收到可疑訊息可以直接貼給 AI 問問看「這是不是詐騙」。
第三點是這頁的翻轉。前兩點都是防守,第三點把 AI 變成幫手:對於不好意思一直打電話問子女的長輩,有一個隨時可以問、不會不耐煩的對象,其實是很實際的防詐工具。詐騙話術相當固定,急迫感、要求保密、指定匯款方式,這些模式 AI 抓得出來,而且不會像家人一樣問「怎麼又點了」。
收尾那句「AI 是很好的防詐諮詢對象,但別讓自己的資料變成詐騙的素材來源」,是這二十六頁裡我最想讓對方記住的一句。如果整場只能留下一句話,我希望是這句。
簡報要好看,不然長輩看兩頁就覺得複雜;也要能在客廳電視上直接播,不然做再漂亮都是零。所以兩種格式都做:一份設計稿負責視覺與線上翻閱,一份 PowerPoint 負責播放。為了避免兩邊各走各的,二十六頁的文字、編號、配色與版型規則全部收斂成單一份內容來源,兩種輸出都從它產生。
過程中有兩道檢查值得記下來。
第一道是內容檢查。二十六頁自己看很難看出問題,改成換一份沒有前後文的視角重看一遍,它不知道我想寫什麼,只看到頁面上實際有什麼,反而抓得到。跟程式的 code review 是同一件事:驗證不能自己驗自己。
第二道是去 AI 味。整份逐行掃過,抓到的唯一一種痕跡是破折號被過度使用,十一處用「——」把兩句話黏成一句。
為了把「AI 為什麼會這樣回答」講成一句白話,我得先把自己的理解壓縮到能用一句話說完,壓不下去的,通常代表我也只是熟悉術語而不是真的懂。
明天是最後一天,會回頭檢視這三十天最初提出的分工假說,看看三個介面各自的邊界是不是站得住腳。
Anthropic 官方文件
其他 AI 平台
模型評比與排行
本篇產出
註一:文中的模型版本、產品功能與介面描述以 2026 年 9 月為準。AI 產品迭代很快,實際操作前請以各家官方最新說明為準。
註二:簡報中的保健食品範例,僅用於示範 AI 生成 Office 檔案的能力,不構成醫療、藥事或營養建議。實際服用種類、劑量與交互作用,請諮詢醫師或藥師。
註三:對中國模型的使用建議,屬於個人在資料落地與內容審查上的考量;各服務的實際條款請以其官方說明為準。
註四:本篇的簡報內容與排版皆為單次製作的結果,屬定性紀錄而非統計證據。
註五:文中提及的 Gemini Notebook 相關功能(知識庫、影片轉逐字稿、Audio Overview)以撰稿當下的公開資訊為準,功能名稱與可用範圍可能已調整。